
Log Dosyaları: AI Arama Stratejisinin Görmezden Gelinen Verisi
Teknik SEO denetimlerinde en sık atlanan dosya, en çok bilgi taşıyan dosya oluyor. Sunucu logları, sitenizde kimin ne zaman ne istediğini satır satır kaydediyor — ve 2026’da bu kayıtların içinde yeni bir grup var: yapay zekâ tarayıcıları.
Content Marketing Institute’un Conductor ile yürüttüğü çalışma basit ama önemli bir örüntüye işaret ediyor: bir AI botunun belirli sayfalara tekrar tekrar dönmesi ile o sayfaların AI cevaplarında kaynak gösterilmesi arasında görünür bir ilişki var. Yani log verisi, görünürlüğün öncü göstergesi olabiliyor. Diğer teknik SEO içerikleri için ana sayfaya bakabilirsiniz.
İçindekiler
- Log Dosyası Aslında Neyi Kaydediyor?
- AI Botları Neden Önemli Bir Sinyal?
- Adım Adım Log Analizi
- Taranmayan Sayfalarla Ne Yapmalı?
- robots.txt ve CDN Tarafındaki Tuzaklar
- Aylık Rutine Dönüştürmek
- Sıkça Sorulan Sorular

Log Dosyası Aslında Neyi Kaydediyor?
Her istek için sunucunuz birkaç bilgi yazıyor: isteği yapanın IP adresi, kendini nasıl tanıttığı (user agent), hangi adresi istediği, ne zaman istediği ve sunucunun hangi yanıt kodunu verdiği.
Analitik araçlarından farkı burada. Google Analytics ya da benzeri araçlar JavaScript ile çalıştığı için botları büyük ölçüde görmüyor. Search Console yalnızca Google’ın kendi tarayıcısını gösteriyor. Log dosyası ise ayrım yapmadan hepsini kaydediyor — arama motoru botları, AI tarayıcıları, kötü niyetli tarayıcılar, hepsi orada.
Yani AI botlarının davranışını görebileceğiniz pratikte tek yer burası.
AI Botları Neden Önemli Bir Sinyal?
Bir sayfanın AI cevaplarında kaynak gösterilebilmesi için önce o sayfanın alınmış ve işlenmiş olması gerekiyor. Tarama, atıfın ön şartı.
Log verisinde takip etmeye değer başlıca tarayıcılar şunlar: GPTBot, Google-Extended, ClaudeBot, PerplexityBot ve son dönemde artan diğer sağlayıcı botları. Bunların ziyaret sıklığı ve hangi sayfalara yoğunlaştığı, içerik stratejinizin AI tarafında nasıl karşılık bulduğunu gösteriyor.
Dikkat edilmesi gereken üç örüntü var:
Tekrar eden ziyaretler. Aynı sayfaya düzenli dönüş, o içeriğin değerli bulunduğunun işareti. Bu sayfaların güncelliğini korumak öncelikli hâle geliyor.
Hiç ziyaret edilmeyen bölümler. Site haritanızda olup log’da hiç görünmeyen sayfalar, AI tarafında pratikte yok hükmünde.
Hata kodu alan istekler. Botun istediği ama 404 ya da 5xx dönen adresler, hem tarama bütçesi israfı hem de içerik kaybı demek. Bot trafiğinin genel yükselişi konusunu 2027’de Bot Trafiği İnsan Trafiğini Geçecek yazısında ele almıştım.
Adım Adım Log Analizi
1. Dosyaya erişin. Paylaşımlı hostingde kontrol panelindeki “raw access logs” bölümünden, kendi sunucunuzda genelde /var/log/nginx/access.log ya da Apache karşılığından, CDN kullanıyorsanız sağlayıcının log dışa aktarma özelliğinden alabiliyorsunuz. CDN kullanıyorsanız asıl kaynak orası — çünkü istekler sunucuya hiç ulaşmadan önbellekten dönüyor olabilir.
2. AI botlarını filtreleyin. User agent alanında bot isimlerini arayın. Basit bir komutla başlayabilirsiniz; tabloya aktarıp bot bazında saymak ilk turda yeterli oluyor.
3. En çok taranan yirmi adresi çıkarın. Bu liste, sitenizin AI gözündeki “önemli sayfalar” listesi. Kendi düşündüğünüz önemli sayfa listesiyle karşılaştırın — arada fark varsa, orası üzerinde çalışılacak yer.
4. Yanıt kodlarını gruplayın. 200 dışındaki her kod bir soru işareti. Özellikle bot isteklerinde yoğun 404 görüyorsanız, silinmiş ama hâlâ dış bağlantı alan sayfalarınız var demektir; bunları yönlendirmek hızlı bir kazanç.
5. Zaman içindeki değişimi izleyin. Tek seferlik bir bakış az şey söylüyor. Asıl değer, yeni içerik yayınladıktan sonra tarama davranışının nasıl değiştiğini görmekte.
Taranmayan Sayfalarla Ne Yapmalı?
Bir sayfa hiç taranmıyorsa sebebi genelde şu dört başlıktan biri oluyor.
Erişim engeli. robots.txt ya da sunucu seviyesinde bir kural botu engelliyor olabilir. En sık karşılaşılan ve en kolay çözülen sebep bu.
İç bağlantı yokluğu. Siteniz içinde hiçbir yerden link almayan sayfa, bot tarafından zor keşfediliyor. Site haritasında olması yeterli değil; gerçek bir sayfadan link alması gerekiyor.
JavaScript bağımlılığı. İçerik yalnızca tarayıcıda çalışan kodla oluşuyorsa, birçok AI tarayıcısı bunu göremiyor. Sunucu tarafında da anlamlı bir HTML dönmesi gerekiyor.
İnce içerik. Yüz kelimelik, özgün bilgi taşımayan sayfalar taranmaya değer bulunmuyor. Bu durumda çözüm sayfayı iyileştirmek ya da birleştirmek.
robots.txt ve CDN Tarafındaki Tuzaklar
Bu bölümü özellikle ayırıyorum, çünkü sahada en çok buradan hata çıkıyor.
Birincisi, CDN sağlayıcıları AI botlarına yönelik varsayılan engelleme politikaları uygulayabiliyor. Ayar panelinde açıkça izin vermediğiniz sürece, siz farkında olmadan tüm AI trafiğini kesiyor olabilirsiniz. Log’da hiç AI botu görmüyorsanız ilk bakılacak yer burası.
İkincisi, robots.txt’te geçmişte iyi niyetle eklenmiş engelleme satırları. Birkaç yıl önce “içeriğim eğitim verisi olmasın” diye eklenen kurallar, bugün AI aramada görünmeme sonucunu doğuruyor olabilir. Bu bilinçli bir tercihse sorun yok; unutulmuş bir satırsa maliyeti yüksek.
Üçüncüsü, sahte bot trafiği. Kendini GPTBot olarak tanıtan ama gerçekte olmayan istekler var. Ciddi bir analiz yapacaksanız IP doğrulaması yapmak gerekiyor; aksi hâlde tarama sayılarını olduğundan yüksek görürsünüz.
Bu tarafla ilgili teknik denetim yaklaşımını SEO Vaka Çalışması: 6 Teknik Düzeltme yazısında somut örneklerle anlatmıştım.
Aylık Rutine Dönüştürmek
Tek seferlik analiz merak giderir, rutin analiz strateji üretir. Ayda bir saatlik bir kontrol yeterli:
Bot bazında toplam istek sayısı geçen aya göre nasıl değişti? Yeni yayınlanan içerikler taranmaya başladı mı, kaç günde? Hangi içerik türü daha sık taranıyor — tanım içerenler mi, liste formatındakiler mi, veri içerenler mi? Hata kodu alan istek sayısı arttı mı?
Bu dört sorunun cevabını bir tabloda biriktirdiğinizde, altı ay sonra elinizde içerik kararlarını gerçekten yönlendirebilecek bir veri seti oluyor. Diğer teknik yazılar için SEO kategorisine göz atabilirsiniz.
Sıkça Sorulan Sorular
Log dosyasına erişimim yok, ne yapabilirim?
Hosting sağlayıcınızdan talep edin; çoğu durumda panelde kapalı gelen bir özellik olarak duruyor. CDN kullanıyorsanız log dışa aktarma genelde daha üst paketlerde açılıyor. Hiçbiri mümkün değilse, sunucu tarafında basit bir erişim kaydı tutan hafif bir çözüm kurmak da bir seçenek.
AI botlarını engellemeli miyim?
Bu bir strateji tercihi. İçeriğinizin AI cevaplarında görünmesini istiyorsanız engellemeyin. İçeriğiniz ücretli bir ürünün parçasıysa ya da özgün araştırma verisi barındırıyorsa engellemek savunulabilir. Kararı verirken şunu göz önünde tutun: engelleme, hem eğitim verisi olmayı hem de cevaplarda kaynak gösterilmeyi birlikte kapatıyor.
Ne kadar geriye dönük log saklamalıyım?
Üç ay çoğu analiz için yeterli, altı ay ideal. Sürekli saklamak disk maliyeti yaratıyor; ayrıca log dosyaları IP adresi içerdiği için KVKK kapsamında kişisel veri sayılabiliyor. Saklama süresini belirleyip aydınlatma metninize yazmak doğru yaklaşım.
Küçük bir sitede bu analiz zahmete değer mi?
Küçük sitede daha da değerli olabiliyor, çünkü sayfa sayısı az olduğu için hangi sayfanın taranıp taranmadığını tek bakışta görüyorsunuz. Yüz sayfalık bir sitede on sayfanın hiç taranmadığını fark etmek, o on sayfayı hızlıca düzeltmek anlamına geliyor.
Tarama sıklığı arttıysa görünürlük de artmış mıdır?
Doğrudan bir garanti değil, ama olumlu bir öncü gösterge. Tarama, atıfın ön şartı olduğu için taranmayan sayfanın görünme ihtimali yok. Yine de asıl doğrulama, ilgili sorguları AI araçlarında elle test edip markanızın geçip geçmediğine bakmakla yapılıyor.
Aklınızda Kalsın
AI görünürlüğü konusunda çoğu ekip tahminle çalışıyor. Oysa sunucunuz aylardır bu sorunun cevabını kaydediyor.
Bu hafta yapılacak iş basit: son otuz günün log dosyasını indirin, AI bot isteklerini filtreleyin ve en çok taranan on sayfayı listeleyin. O liste, sizin AI tarafındaki gerçek içerik envanteriniz. Beklediğinizden farklı çıkarsa, strateji tartışması oradan başlıyor.
Teknik tarafta destek isterseniz SEO & SEM danışmanlığı sayfasından iletişime geçebilirsiniz.
Kaynakça
Content Marketing Institute. (2026, Mart). Try this underused tactic to get your content cited in AI search. https://contentmarketinginstitute.com/generative-engine-optimization/content-cited-in-ai-search
Search Engine Journal. (2026). Ask an SEO: Should SEOs use log file data? https://www.searchenginejournal.com/ask-an-seo-should-seos-use-log-file-data/567932/
Hasan Yasin TÜRKYILMAZ sitesinden daha fazla şey keşfedin
Subscribe to get the latest posts sent to your email.


